TD
The Decoder • 43일 전
IMP 7
러시아 선전에 속는 AI 모델들, 에스토니아 연구소가 실험하다
에스토니아어 연구소가 AI 언어 모델이 러시아 선전에 얼마나 취약한지 평가하는 새로운 벤치마크를 발표했습니다. 테스트 결과 앤스로픽의 클로드(Claude) 모델이 가장 우수한 성능을 보인 반면, 유럽의 대안을 표방하는 프랑스 기업 미스트랄(Mistral)의 모델은 가짜 뉴스를 걸러내는 데 가장 취약한 것으로 나타났습니다. 이는 악의적인 외국 세력이 AI를 허위 정보 유포에 악용하는 보안 위협이 현존하며, 모델별 대응 능력 편차가 큼을 시사합니다.
AI 안전 가짜 뉴스 벤치마크